PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

Fang, Jiarui; Pan, Jinzhe; Wang, Jiannan; Li, Aoyu; Sun, Xibo

Computer Science > Computer Vision and Pattern Recognition

arXiv:2405.14430 (cs)

[Submitted on 23 May 2024 (v1), last revised 31 Oct 2024 (this version, v3)]

Title:PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

Authors:Jiarui Fang, Jinzhe Pan, Jiannan Wang, Aoyu Li, Xibo Sun

View PDF HTML (experimental)

Abstract:This paper presents PipeFusion, an innovative parallel methodology to tackle the high latency issues associated with generating high-resolution images using diffusion transformers (DiTs) models. PipeFusion partitions images into patches and the model layers across multiple GPUs. It employs a patch-level pipeline parallel strategy to orchestrate communication and computation efficiently. By capitalizing on the high similarity between inputs from successive diffusion steps, PipeFusion reuses one-step stale feature maps to provide context for the current pipeline step. This approach notably reduces communication costs compared to existing DiTs inference parallelism, including tensor parallel, sequence parallel and DistriFusion. PipeFusion also exhibits superior memory efficiency, because it can distribute model parameters across multiple devices, making it more suitable for DiTs with large parameter sizes, such as Flux.1. Experimental results demonstrate that PipeFusion achieves state-of-the-art performance on 8xL40 PCIe GPUs for Pixart, Stable-Diffusion 3 and Flux.1 this http URL Source code is available at this https URL.

Subjects:	Computer Vision and Pattern Recognition (cs.CV); Artificial Intelligence (cs.AI); Performance (cs.PF)
Cite as:	arXiv:2405.14430 [cs.CV]
	(or arXiv:2405.14430v3 [cs.CV] for this version)
	https://doi.org/10.48550/arXiv.2405.14430

Submission history

From: Jiarui Fang [view email]
[v1] Thu, 23 May 2024 11:00:07 UTC (24,855 KB)
[v2] Sun, 26 May 2024 04:57:33 UTC (10,866 KB)
[v3] Thu, 31 Oct 2024 05:14:31 UTC (14,609 KB)

Computer Science > Computer Vision and Pattern Recognition

Title:PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

Submission history

Access Paper:

References & Citations

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators

Computer Science > Computer Vision and Pattern Recognition

Title:PipeFusion: Patch-level Pipeline Parallelism for Diffusion Transformers Inference

Submission history

Access Paper:

References & Citations

BibTeX formatted citation

Bookmark

Bibliographic and Citation Tools

Code, Data and Media Associated with this Article

Demos

Recommenders and Search Tools

arXivLabs: experimental projects with community collaborators